AI资讯新闻榜单内容搜索- DeepSeek

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索:  DeepSeek
偷偷分享 DeepSeek Harness 热榜挖到的 2 个实⽤插件

偷偷分享 DeepSeek Harness 热榜挖到的 2 个实⽤插件

偷偷分享 DeepSeek Harness 热榜挖到的 2 个实⽤插件

太猛了,DeepSeek Harness 截至当前已经 112 k 的 Star 了,而这距发布仅仅过去三天。而且还在以惊人的速度增长...DeepSeek Harness 的核心就是:一切皆插件。说个不确切的比喻,有点 Agent 时代的 Obsidian 感觉了,自由度太高了。

来自主题: AI资讯
8323 点击    2026-08-16 21:58
梁神变牢梁的原因找到了!疑似 DeepSeek 发错模型,HF配置和API后台紧急切换

梁神变牢梁的原因找到了!疑似 DeepSeek 发错模型,HF配置和API后台紧急切换

梁神变牢梁的原因找到了!疑似 DeepSeek 发错模型,HF配置和API后台紧急切换

DeepSeek-v4-pro-0813 正式上线,两极分化的口碑却让人摸不着头脑。一边,是疯狂刷屏的评测夯爆了:多项 Agent 测试逼近 Fable 5,被认为是又一次前沿模型的“核弹级”更新;另一边,却是不少深夜忠实开发者直摇头:吐槽涨价、模型能力不及预期,实测体感甚至不如之前的小模型……

来自主题: AI资讯
8430 点击    2026-08-16 21:33
刚刚,DeepSeek Harness震撼开源:一切皆插件

刚刚,DeepSeek Harness震撼开源:一切皆插件

刚刚,DeepSeek Harness震撼开源:一切皆插件

今天凌晨,DeepSeek V4 Pro 正式版发布,引发热潮。现在,半天过去,DeepSeek Harness (开发者预览版)也来了!当然,这并不意外,毕竟该项目之前已经铺垫了很久了,比如 DeepSeek Harness 团队的崔添翼就一直在社交网络上发预热贴以及为该团队招募人才。

来自主题: AI资讯
10544 点击    2026-08-14 00:23
突发 | DeepSeek V4 Pro 上线,逼近 Fable 5

突发 | DeepSeek V4 Pro 上线,逼近 Fable 5

突发 | DeepSeek V4 Pro 上线,逼近 Fable 5

就在刚刚,DeepSeek V4 Pro 正式版来了。最新的模型与价格页面显示,deepseek-v4-pro 对应模型版本已经更新为 DeepSeek-V4-Pro-0813。从目前公布的信息来看,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。

来自主题: AI资讯
9525 点击    2026-08-13 00:03
给 Codex 和 Claude Code 接入 DeepSeek-V4-Flash,夯爆了!

给 Codex 和 Claude Code 接入 DeepSeek-V4-Flash,夯爆了!

给 Codex 和 Claude Code 接入 DeepSeek-V4-Flash,夯爆了!

其实 Codex 和 Claude Code 都支持切换模型,咱们直接用 DeepSeek-V4-Flash 来驱动它们就行,量大管饱、不用魔法、也不怕封号。而且现在 DeepSeek 官方已经做了原生适配,接入流程比以前简单多了。

来自主题: AI资讯
9769 点击    2026-08-03 16:14
实习生日薪 5500 元,清华姚班凭什么成为 AI 圈的「硬通货」

实习生日薪 5500 元,清华姚班凭什么成为 AI 圈的「硬通货」

实习生日薪 5500 元,清华姚班凭什么成为 AI 圈的「硬通货」

最近,DeepSeek 接连上了几次热搜。先是因为一张实习 offer 引发围观。一位清华学生在社交媒体晒出录用信息,岗位是 DeepSeek 实习生,税前日薪 5500 元。按每月 22 个工作日计算,月薪超过 12 万元。

来自主题: AI资讯
9299 点击    2026-07-25 21:16
梁文锋四小时投资人会议实录

梁文锋四小时投资人会议实录

梁文锋四小时投资人会议实录

@elsewhere 上个月,「elsewhere」报道了 DeepSeek 的融资故事。其中最多人讨论的,莫过于那个传说中的4小时投资人会议。 此去一个月间,梁文锋的各种语录在江湖流传,我们也多方收集到了一些其中内容。

来自主题: AI资讯
9929 点击    2026-07-23 09:22
让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

随着 DeepSeek 发布 DSpark,动态 MTP(多 Token 预测)成为了对抗高并发、提升 GPU 利用率的绝对焦点。然而,DSpark 高度绑定特定模型且需要额外训练。

来自主题: AI技术研报
9394 点击    2026-07-17 10:08
ISSTA 2026|LAVE:面向扩散语言模型的约束解码

ISSTA 2026|LAVE:面向扩散语言模型的约束解码

ISSTA 2026|LAVE:面向扩散语言模型的约束解码

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

来自主题: AI技术研报
9204 点击    2026-07-16 10:09
用推理步骤的「语义冗余」给LRM过度思考踩刹车

用推理步骤的「语义冗余」给LRM过度思考踩刹车

用推理步骤的「语义冗余」给LRM过度思考踩刹车

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

来自主题: AI技术研报
6042 点击    2026-07-16 10:08